
Gemini 4
Découvrez l'API Gemini 4.

Découvrez l'API Gemini 4.

Gemini 3.8 Flash est un modèle Gemini léger de nouvelle génération, ayant pour objectif d’atteindre un meilleur équilibre entre la vitesse, le coût et les capacités de codage.

Le modèle Gemini 3.1 Flash Lite Image est un spécialiste de l’efficacité au sein de la famille de modèles de génération d’images, conçu pour une latence ultra-faible et pour une génération et une modification d’images à moindre coût.

Gemini 3.5 Flash est un modèle d’IA à grande vitesse, conçu pour une réponse rapide et des performances de codage efficaces. Il offre une vitesse de génération nettement améliorée tout en conservant de solides capacités de raisonnement, ce qui le rend adapté aux applications en temps réel et aux flux de travail des développeurs.

3.7 Flash apporte des améliorations significatives dans les flux de travail de l’ingénierie logicielle, du travail intellectuel et du développement web — avec un prix de lancement équivalent à la moitié du coût initial de 3.6 Flash par million de jetons.

Gemini 3.1 Pro est la prochaine génération dans la série de modèles Gemini, une suite de modèles de raisonnement hautement performants, nativement multimodaux. Gemini 3 Pro est désormais le modèle le plus avancé de Google pour les tâches complexes, et peut comprendre de vastes ensembles de données ainsi que des problèmes difficiles issus de différentes sources d’information, y compris le texte, l’audio, les images, la vidéo et des dépôts de code entiers.

Gemini 3.6 Flash offre une intelligence de pointe soutenue, optimisée pour des tâches du monde réel, à une vitesse supérieure et à moindre coût. Conçu pour l’ère agentique, il excelle en génération de code, en exécution agentique et en raisonnement spatial. Ce modèle est particulièrement efficace pour des boucles agentiques rapides impliquant des cycles et des itérations de codage complexes.

Aperçu des capacités principales: Résolution: Jusqu'à 4K (4096×4096), comparable à Pro. Cohérence des images de référence: Jusqu'à 14 images de référence (10 objets + 4 personnages), en maintenant la cohérence du style et des personnages. Rapports d'aspect extrêmes: Nouveaux rapports 1:4, 4:1, 1:8, 8:1 ajoutés, adaptés aux images longues, aux affiches et aux bannières. Rendu de texte: Génération de texte avancée, adaptée aux infographies et aux mises en page d'affiches marketing. Amélioration de la recherche: Google Search + Image Search intégrés. Ancrage: Processus de réflexion intégré; les prompts complexes font l'objet d'un raisonnement avant la génération.

Gemini Omni Fast est un modèle multimodal léger de génération vidéo, conçu pour une création de contenu rapide et flexible. Il permet une génération vidéo efficace grâce à la prise en charge de plusieurs types d’entrée, ce qui le rend adapté aux flux de travail interactifs et itératifs.
Veo 3.1 Fast est une version optimisée de Veo 3.1 conçue pour la génération rapide de vidéos et une production à haut débit. Elle conserve une qualité visuelle élevée tout en améliorant considérablement la rapidité, ce qui la rend adaptée à la création de contenus par lots et à des flux de travail évolutifs.

Veo 3.1 est un modèle phare de génération vidéo par IA, conçu pour un rendu cinématographique de haute qualité avec une synchronisation audio native. Il offre des mouvements réalistes, une grande fidélité visuelle et une génération audio-visuelle étroitement synchronisée pour la production vidéo professionnelle.

Gemini 3.1 Flash-Lite est un modèle Tier-3 très économique et à faible latence de la série Gemini 3 de Google, conçu pour des flux de travail d’IA en production à fort volume où le débit et la vitesse priment sur la profondeur de raisonnement maximale. Il combine une vaste fenêtre de contexte multimodale et des performances d’inférence efficaces, à un coût inférieur à celui de la plupart des modèles phares.

Nano Banana Pro est un modèle d’IA destiné à fournir une assistance polyvalente dans des flux de travail centrés sur le texte. Il convient aux prompts de type instruction pour générer, transformer et analyser du contenu avec une structure contrôlable. Les cas d’utilisation typiques incluent les assistants de chat, la synthèse de documents, la question-réponse (QA) basée sur les connaissances et l’automatisation des flux de travail. Les détails techniques publics sont limités ; l’intégration s’aligne sur les schémas courants des assistants d’IA, tels que les sorties structurées, les prompts augmentés par la recherche et l’appel d’outils ou de fonctions.
Veo 3 Fast est la variante de la famille Veo de modèles vidéo génératifs de Google, optimisée pour la vitesse (Veo 3 / Veo 3.1, etc.). Il est conçu pour produire de courts clips vidéo de haute qualité avec une piste audio générée nativement, tout en privilégiant le débit et le coût par seconde — en sacrifiant une partie de la fidélité visuelle haut de gamme et/ou des durées de plan plus longues au profit d’une génération beaucoup plus rapide et d’un coût inférieur. Qu’est-ce que Veo 3 Fast — présentation concise
Veo 3 de Google DeepMind représente l’état de l’art de la génération de vidéo à partir de texte, marquant la première fois qu’un modèle d’IA générative à grande échelle synchronise de manière transparente une vidéo haute fidélité avec l’audio qui l’accompagne — y compris les dialogues, les effets sonores et les ambiances sonores.

Gemini 3 Flash est un modèle multimodal à grande échelle, léger et efficace, de Google, conçu pour des cas d’usage réels nécessitant des réponses rapides et une faible latence.
gemini-3.1-flash bientôt disponible

à venir
Gemini 3.5 Flash-Lite est un modèle multimodal à faible latence et économique, optimisé pour une exécution à haut débit et à faible coût pour des tâches de sous-agents et l’analyse de documents. Le modèle prend en charge des entrées texte, image, vidéo, audio et PDF, et est conçu pour des flux de travail basés sur des agents à grande échelle, l’extraction simple de données et des applications où la latence et le coût de l’API sont les principales contraintes.

Bientôt disponible